📝 Резюме · 🧾 Транскрипт (формат) · 📄 Оригинал (3.0 KB)
https://t.me/SberAIScience/4309

ИИ, который оказался слишком сильным для рынка

Источник: https://t.me/SberAIScience/4309

Краткое содержание

9 июня 2026 года Anthropic выпустила две модели: Claude Mythos 5 и Claude Fable 5. По сути это одна и та же LLM, но Fable 5 дополнительно обёрнута в более жёсткие классификаторы безопасности. Через три дня доступ к обеим моделям был закрыт по запросу правительства США, сославшегося на угрозу национальной безопасности.

Ключевые возможности моделей

  • Большой контекст — генерация ответов до 128 тысяч слов; работа с крупными файлами и архивами, опора на собственные заметки в процессе рассуждений
  • Инженерные задачи — разбор масштабных кодовых баз; по заявлениям разработчиков, способна за один день выполнить миграцию проекта объёмом десятки миллионов строк кода
  • Визуальный анализ — извлечение точных значений из научных графиков, восстановление кода веб-приложения по скриншотам
  • Научные задачи — ускорение дизайна белков для лекарств примерно в 10 раз; автономная работа в геномике на протяжении нескольких дней с минимальным участием человека

Результаты на бенчмарках

Fable 5 установила рекорд на SWE-bench Verified — 95% решённых задач против прежнего рекорда 88,6% (Opus 4.8). Задания бенчмарка предполагают анализ реальных кодовых баз из GitHub и исправление ошибок.

Значимость

Запрет со стороны правительства США стал, по иронии, самым громким подтверждением возможностей модели. Инцидент поднимает вопрос о том, где проходит граница между коммерческим ИИ-инструментом и технологией, требующей государственного регулирования.

🧾 Транскрипт (формат)

ИИ, который оказался слишком сильным для рынка 🤩

Источник: https://t.me/SberAIScience/4309

ИИ, который оказался слишком сильным для рынка 🤩

9 июня Anthropic запустила на рынок Claude Mythos 5 и Claude Fable 5. По сути, это одна и та же LLM, но Fable 5 дополнительно обёрнута в более жёсткие классификаторы безопасности.

А через три дня доступ к ним пришлось отключить 🤩

Компания сделала это по просьбе правительства США, которое сослалось на угрозу национальной безопасности. И это, пожалуй, самый громкий комплимент возможностям Claude.

Почему вокруг модели столько шума? 🤩 🟣 Умеет долго держать огромный контекст Работает с большими файлами, архивами и материалами. Генерирует ответы до 128 тысяч слов, а также умеет опираться на свои же заметки

🟣 Решает инженерные задачи уровня большой команды Разбирает крупные кодовые базы и, по заявлениям разработчиков, может справляться с миграцией проекта на десятки миллионов строк кода за день

🟣 Работает с визуальными данными Достаёт точные значения из научных графиков, анализирует изображения и может восстанавливать код веб-приложения по скриншотам

🟣 Ускоряет сложную научную работу В задачах по дизайну белков для лекарств даёт прирост скорости примерно в 10 раз, а в геномике способна несколько дней работать почти без участия человека

Fable 5 уже поставила рекорд на SWE-bench Verified — бенчмарке, где модели анализируют кодовые базы из GitHub и исправляют ошибки. 95% решённых задач против 88,6% у прежнего лидера Opus 4.8. Хотя самым важным бенчмарком всё-таки стал её запрет 🤩

Для чего использовали бы такой ИИ? ❤️ — сделал бы задачи на месяц вперёд 🤔 — наконец выяснил, чего хочет принтер

✔️ Подписывайтесь на Sber AI в МАКС